Objetivos de Aprendizagem
- Descrever o ciclo de vida de pré-treinamento e ajuste fino dos LLMs.
- Explorar o aprendizado por reforço a partir de feedback humano (RLHF).
- Praticar engenharia de prompts e métodos de ajuste fino com eficiência de parâmetros (PEFT/LoRA).